메뉴

#모드 붕괴

TD
The Decoder • 36일 전
IMP 6

AI 텍스트 탐지가 가능한 이유: 안전장치가 좁히는 표현 범위

AI 텍스트 탐지 업체 팡그램(Pangram)의 CTO 브래들리 에미는 LLM이 이론상 인간처럼 다양하게 쓸 수 있지만, 후 훈련(post-training)과 안전 가드레일이 표현 범위를 좁혀 '모드 붕괴(mode collapse)'를 유발해 텍스트가 탐지 가능해진다고 주장했습니다. 후 훈련 전 기반 모델이나 특정 작가·특정 커뮤니티에만 파인튜닝된 모델은 탐지되지 않지만, 워터마크가 삽입된 텍스트는 항상 탐지 가능하다는 점이 핵심입니다.

AI 텍스트 탐지 LLM 안전성
40
404 Media • 107일 전
IMP 7

AI 챗봇이 '등대지기 일라이어스'를 반복하는 이유

최근 주요 AI 챗봇들에게 이야기를 creation(생성)하라고 하면 '등대지기 일라이어스 쏜(Elias Thorne)'이라는 허구의 인물이 88% 이상 빈번하게 등장하는 현상이 발견되었습니다. 코넬 대학교 연구진에 따르면, 이는 OpenAI의 초기 데이터셋에서 시작된 특정 문체가 다른 모델들의 학습 과정에서 마치 바이러스처럼 복제되었기 때문입니다. 결국 이 이름은 챗봇을 벗어나 아마존의 가짜 AI 저서나 유튜브 영상 등에 무분별하게 사용되며 디지털 생태계를 오염시키는 핵심 사례로 지목되고 있습니다.

AI 환각 현상 대형 언어 모델 학습 데이터 오염